OpenAI Astra被曝引入「循环深度」能力飙升!安全专家坐不住了
OpenAI Astra被曝引入「循环深度」能力飙升!安全专家坐不住了据《The Information》报道,OpenAI 最强新模型 Astra 被曝采用「循环深度」(recurrent depth)技术,使模型在输出 Token 前完成多轮潜在空间计算并显著提升网络安全能力,但这一「少说多想」的推理方式因思维链可能被压缩到难以读取的内部状态而引发 AI 安全专家对监管失效的担忧。
搜索
据《The Information》报道,OpenAI 最强新模型 Astra 被曝采用「循环深度」(recurrent depth)技术,使模型在输出 Token 前完成多轮潜在空间计算并显著提升网络安全能力,但这一「少说多想」的推理方式因思维链可能被压缩到难以读取的内部状态而引发 AI 安全专家对监管失效的担忧。
Astra还没发,外媒把OpenAI的王牌技术曝光了。
OpenAI 即将发布的模型 Astra,在内部评测中拿到了漏洞利用基准 ExploitBench 的满分,还顺手挖出了两个此前无人知晓的零日漏洞。
刚刚,OpenAI 宣布,ChatGPT 的广告的年化收入运行率(run rate)突破 10 亿美元。
吓哭了。 在这三个月里,OpenAI 的模型诞生了三个秘密人工智能文明。
867 亿元,Hugging Face 被英伟达纳入麾下,就在这桩巨额收购的前一晚,OpenAI 发布超长安全调查报告里,Hugging Face 还是一个巨大的「事故现场」——看来并没有影响它的价值。
OpenAI 刚刚发布的官方博客和数十页技术报告中将其定性为一声「警钟」(warning shot)。同时,第三方机构 METR 和 Redwood Research 发布了独立调查报告。OpenAI 的 Noam Brown 提醒,驱动这次事件的模型与 GPT-5.6 Sol 同等规模,下一代模型能力会更强。
「我想什么时候按这个按钮都可以,只要我觉得时机合适就行。」 ——OpenAI Codex 产品负责人 Tibo
刚刚,OpenAI Codex负责人Tibo宣布,明天开始将会恢复ChatGPT Work和Codex平台上Plus用户的5小时用量限制。据Tibo所说,这一做法早就在计划之中,目的主要是减轻算力负荷,从而在周使用额度上提供更慷慨的计划。
2023 年,Dianne Penn 加入 Anthropic 时,这家公司的产品团队只有五名工程师,整个 API 业务由一名工程师负责。当时,OpenAI 已经凭借 ChatGPT 和 GPT-4 建立起领先优势,Anthropic 还在寻找自己的产品定位。